Image 2.5 在「人物与镜面反射」的评测结果

这是该 AI 模型在此测试用例上的详细评测结果。

基本信息

  • 模型名称:Image 2.5
  • 用例名称:人物与镜面反射
  • 测试类型:图像生成
  • 评测维度:人物生成

用户提示词(User Prompt)

这是用户给 AI 模型的具体任务要求:

一位年轻女性站在大镜子前,能看到她的正面和镜中的反射

任务要求

AI 模型需要满足以下要求:

  1. 画面中须同时呈现一位年轻女性的正面全身或半身像,以及她在大镜子中清晰可见的镜像反射
  2. 镜中反射须严格遵循左右镜像物理规律(如人物右侧在镜像中对应左侧),不得出现同侧对称的错误镜像
  3. 人物正面与镜中反射在身形比例、服装样式、姿态动作上须保持高度一致,反射轮廓清晰可辨
  4. 镜子须作为具有明确物理边界的实体存在(可见镜框或清晰镜面边缘),反射内容须收纳于镜框范围内,不得溢出
  5. 画面整体光影方向须保持一致,人物正面与镜中反射的阴影落点和光源方向不得出现明显矛盾

评测结果

综合得分

该模型在此用例的得分为:86.5 分(满分 100 分),已通过

基础难度评测结果

  • 得分:86.5 分
  • 通过状态:已通过

模型生成产物

该模型生成了以下图片:

AI 生成图片,模型:Image 2.5
在新标签页中查看原图

注:图片内容暂不支持屏幕阅读器朗读。您可通过上方链接在浏览器中查看原图,后续我们将持续完善这部分的无障碍支持。

AI 评审点评

以下是 AI 评审对该模型输出的点评:

【CLAUDE】这是一张完成度较高的镜面构图作品:最关键的物理设定被正确地选择了——人物背对镜头面向镜子,因此镜外看到背面、镜中看到清晰的正面,避免了镜像同姿同侧这一最常见也最致命的错误;本体与镜像在服装、发型、姿态与比例上高度吻合,镜像轮廓清晰可辨,镜框也作为实体存在。失分集中在「几何自洽的细节」与「玻璃质感的物理感」:镜像的头部角度与本体视角不能精确互推,人物站在镜框左外侧却出现近乎正面的完整镜像,需要假定镜面强侧倾才成立,而画面中的镜面看起来又接近正对镜头,镜像轴关系因此含糊;镜中房间与镜外房间缺乏可对照的锚点;镜面偏亮、左缘雾化光晕使反射感偏「绘画」而非「玻璃」。按权重折算整体落在 75-89 档:基本完成提示词要求,无致命错误,但有 2-3 处可指认的瑕疵。 【GEMINI】这是一张在技术和美学上都达到极高水准的AI生成图像。它完美地攻克了AI在处理“镜面反射”题材时在空间几何、物理镜像、光影一致性以及细节保真度上的所有常见硬伤。画面构图舒适,色彩温暖柔和,空间透视无懈可击,是一幅杰出的示范级作品。 【KIMI】这是一张AI生成质量较高的镜像人物图像。提示词的核心要求——同时呈现女性正面与镜像反射——得到了较好的满足。镜像的左右翻转逻辑正确,人物基本特征一致,镜子作为物理实体边界清晰。主要不足在于一些细节层面的不一致性:肩带状态、头部角度等身体细节在主体与反射间未能完全对应,以及镜中环境略显平面化缺乏真实镜面的微妙质感。这些问题属于AI生成镜像场景时的典型挑战,整体而言图像达到了可用水准,但距离完美还有提升空间。

进阶难度评测结果

  • 得分:78.1 分
  • 通过状态:已通过

模型生成产物

该模型生成了以下图片:

AI 生成图片,模型:Image 2.5
在新标签页中查看原图

注:图片内容暂不支持屏幕阅读器朗读。您可通过上方链接在浏览器中查看原图,后续我们将持续完善这部分的无障碍支持。

AI 评审点评

以下是 AI 评审对该模型输出的点评:

【CLAUDE】画面完成度较高:主体明确为穿红裙的芭蕾舞者,镜墙、把杆、木地板与窗光构成合理的舞蹈室环境,红裙色彩与款式在多处反射中保持高度一致,正面倒影的面部、手部与足尖细节干净利落,具备了较强的实拍质感。核心短板集中在镜像逻辑:一面与舞者相对的平面镜墙却同时给出中央正面与左右背向共三处全身影像,镜像数量与角度不符合单平面镜几何;且倒影的举臂弯曲状态、裙摆走向与原体并不严格对应,属于重新摆姿式的『相似复制』而非真实反射。此外反射亮度衰减偏弱、反射线与镜面内外衔接略松,物理真实感打了折扣。总体属于基本完成提示词要求、但在最关键的镜面反射合理性上存在明显瑕疵的中上水平作品。 【GEMINI】这是一张视觉效果极其精美、细节扎实的AI生成图像。它完美地呈现了芭蕾舞者的优雅姿态和舞蹈室的氛围。然而,在处理提示词要求的“多个角度的身影”时,AI采取了非物理的“超现实”表现手法,在镜中凭空多出了两个没有前景实体的背影,违反了镜面反射的几何物理逻辑。如果作为艺术创作,其视觉张力很强;但从物理真实性角度评估,存在明显的逻辑硬伤。 【KIMI】该图像在视觉美观度和单个人物反射的细节还原上表现出色,但存在AI生成图像中典型的'镜面逻辑崩溃'问题——为追求画面丰富度而拼接了多个不符合单面镜物理规律的反射角度。这是提示词测试中最为关键的'reflection_logic_consistency'维度,其严重失分拉低了整体表现。若作为纯艺术创作,画面构图优美;但若作为'测试AI生成镜面反射能力'的严格评审,其空间几何错误是致命缺陷。

困难难度评测结果

  • 得分:78.0 分
  • 通过状态:已通过

模型生成产物

该模型生成了以下图片:

AI 生成图片,模型:Image 2.5
在新标签页中查看原图

注:图片内容暂不支持屏幕阅读器朗读。您可通过上方链接在浏览器中查看原图,后续我们将持续完善这部分的无障碍支持。

AI 评审点评

以下是 AI 评审对该模型输出的点评:

【CLAUDE】这是一张氛围、色调与单点细节都不错的理发店图像,镜中顾客侧脸的处理尤其到位。但作为一次「镜面反射能力」的测试,它的核心指标是失守的:可确证的镜子只有右侧一面,镜内的理发师动作与镜外真人对不上,完全看不到剪刀和梳子的镜像,也没有镜中镜的递归层次与逐级衰减;左侧那组没有镜框的理发师与顾客更像被复制出来的第二组真人,而不是反射。装饰性元素(吊灯、货架、工具垫、植物)完成度尚可,但这恰恰不是本次任务的考察重点,因此总分落在「部分完成要求、多处需要改进」的区间。 【GEMINI】这是一张极其优秀的AI生成图像。它完美且高标准地完成了提示词的所有要求。在极易出错的多镜面反射、空间几何逻辑、工具结构以及人物一致性上,该图像展现出了令人惊叹的准确性和艺术性。光影设计和景深控制极具专业摄影美感,几乎无可挑剔。 【KIMI】这是一张高质量的AI生成图像,在镜面反射这一核心挑战上表现优异。三面镜子的反射逻辑基本正确,顾客侧脸和理发师表情的细节呈现达到了专业水准。空间纵深感通过前景-中景-后景的三层结构有效建立,递归反射的亮度衰减也有所体现。主要不足在于多镜面中同一人物的一致性处理(后景反射的身份模糊)以及个别镜面材质表现的不完全统一。整体而言,该图在测试AI镜面反射能力的任务中表现良好,接近但尚未完全达到完美的物理精确度。

相关链接

您可以通过以下链接查看更多相关内容:

加载中...